6 分钟
TensorFlow 2.0 (九) - 强化学习 70行代码实战 Policy Gradient
TensorFlow2教程,TensorFlow2.0教程,TensorFlow 2.0 入门系列文章,第九篇,使用强化学习算法策略梯度(Policy Gradient),实战 OpenAI gym CartPole,代码仅70行。
TensorFlow2教程,TensorFlow2.0教程,TensorFlow 2.0 入门系列文章,第九篇,使用强化学习算法策略梯度(Policy Gradient),实战 OpenAI gym CartPole,代码仅70行。
TensorFlow2教程,TensorFlow2.0教程,TensorFlow 2.0 入门系列文章,第八篇,强化学习 DQN (Deep Q-Learning) 玩转 OpenAI gym game MountainCar-v0。
TensorFlow2教程,TensorFlow2.0教程,TensorFlow 2.0 入门系列文章,第七篇,Q-Learning 玩转 OpenAI gym game MountainCar-v0。
TensorFlow2教程,TensorFlow2.0教程,TensorFlow 入门系列文章,第六篇,监督学习玩转 OpenAI gym game。